À partir de photos, captures d’écran et PDF scannés, Image en texteet l’OCR PDF sont traités directement sur votre appareil. Les pages PDF avec texte sélectionnable sont lues depuis leur couche de texte au lieu de passer par l’OCR.
JPG, PNG, WebP, BMP, PDF · Les fichiers d'origine ne sont pas envoyés au serveur MISCLAND.
Non. Les images et PDF d'origine que vous sélectionnez ne sont pas envoyés au serveur ; ils sont traités dans la mémoire du navigateur actuel.
Les calculs OCR s'exécutent sur votre PC ou appareil mobile avec PaddleOCR.js et WebAssembly. Le serveur MISCLAND fournit uniquement les fichiers statiques du moteur OCR et des modèles ; il ne reçoit ni ne stocke le contenu des documents ou les résultats OCR.
Si une page PDF contient déjà du texte sélectionnable, PDF.js l'extrait directement. Cette méthode est plus rapide que l'OCR et préserve plus fidèlement le texte d'origine.
Seules les pages numérisées ou les PDF sous forme d'image sans couche de texte sont rendus en images dans votre navigateur puis traités par OCR. Si un PDF contient à la fois des pages texte et des pages numérisées, chaque page est automatiquement traitée avec la méthode appropriée.
Vous pouvez sélectionner le coréen, l'anglais, l'espagnol, le portugais, le français, l'allemand, l'italien, l'indonésien, le vietnamien, l'arabe, l'hindi, le chinois simplifié ou traditionnel et le japonais.
L'outil utilise un modèle mobile de reconnaissance PP-OCRv5 adapté à la langue choisie. Le modèle n'est chargé qu'après sélection de la langue et lancement effectif de l'OCR, puis le cache du navigateur est utilisé lors des exécutions suivantes.
L'OCR ne peut pas garantir une précision de 100 %, car la reconnaissance varie selon la qualité de la source, la taille du texte, l'inclinaison, l'arrière-plan et la police.
Les documents imprimés et les scans nets donnent les meilleurs résultats. Utilisez Haute qualité pour les très petits caractères et essayez Amélioration du document pour les scans noir et blanc peu contrastés. Comparez toujours les résultats importants au document original.
Oui. L'outil fonctionne dans les navigateurs mobiles modernes prenant en charge WebAssembly et les Web Workers.
L'OCR utilise la mémoire et la puissance de calcul de votre appareil ; les appareils modestes ou les documents très volumineux peuvent donc prendre plus de temps. Sur mobile, des limites de sécurité plus basses sont automatiquement appliquées au nombre de fichiers, à la taille totale, aux pages PDF et à la résolution des images.